Noms propres, syntagmes nominaux, expressions référentielles : repérage et codage.
Identifieur interne : 000227 ( France/Analysis ); précédent : 000226; suivant : 000228Noms propres, syntagmes nominaux, expressions référentielles : repérage et codage.
Auteurs : Florence Bruneseaux [France]Source :
Abstract
Parmi les avantages qu'offre la version informatisée d'une ressource linguistique, il y a, entre autres, la possibilité d'enrichir le document d'annotations spécifiques qui ne se limitent pas à un simple repérage de début/fin de sections ou de paragraphes. Dans cet article, nous aborderons plus précisément le problème du repérage et du codage des noms propres, syntagmes nominaux et expressions référentielles. Cependant, si l'annotation des noms propres peut être intéressante à des fins multiples (résumés automatiques, recherche dans des bases de données, etc.), on verra que dans les faits un tel travail suppose une bonne réflexion sur ce que l'on doit effectivement coder. C'est pourquoi, en nous appuyant sur les recommandations de la TEI (Text Encoding Initiative), nous faisons des propositions afin d'aller au-delà des possibilités actuelles et d'offrir ainsi un schéma qui permette d'affiner le codage en fonction du niveau d'analyse auquel le nom propre est appréhendé, distinguant entre nom propre élément d'un syntagme nominal ou d'une expression référentielle. || Among the advantages of an electronic version of a document is the oportunity to include different kinds of annotations which are not restricted to section or paragraph tagging. This paper discusses the encoding of proper names, nominal phrases and referr
Url:
Affiliations:
- France
- Grand Est, Lorraine (région)
- Nancy
- Institut national polytechnique de Lorraine, Université Nancy 2, Université de Lorraine
Links toward previous steps (curation, corpus...)
- to stream Hal, to step Corpus: 000037
- to stream Hal, to step Curation: 000037
- to stream Hal, to step Checkpoint: 000031
- to stream Main, to step Merge: 002603
- to stream Main, to step Curation: 002483
- to stream Main, to step Exploration: 002483
- to stream France, to step Extraction: 000227
Links to Exploration step
Hal:inria-00098462Le document en format XML
<record><TEI><teiHeader><fileDesc><titleStmt><title xml:lang="fr">Noms propres, syntagmes nominaux, expressions référentielles : repérage et codage.</title>
<author><name sortKey="Bruneseaux, Florence" sort="Bruneseaux, Florence" uniqKey="Bruneseaux F" first="Florence" last="Bruneseaux">Florence Bruneseaux</name>
<affiliation wicri:level="1"><hal:affiliation type="researchteam" xml:id="struct-2351" status="OLD"> <idno type="RNSR">199421391G</idno>
<orgName>Human-machine dialogue with a significant language component</orgName>
<orgName type="acronym">LANGUE ET DIALOGUE</orgName>
<desc> <address> <country key="FR"></country>
</address>
</desc>
<listRelation> <relation active="#struct-2496" type="direct"></relation>
<relation active="#struct-300009" type="indirect"></relation>
<relation active="#struct-466633" type="direct"></relation>
<relation active="#struct-300291" type="indirect"></relation>
<relation active="#struct-300292" type="indirect"></relation>
<relation active="#struct-300293" type="indirect"></relation>
<relation name="UMR7503" active="#struct-441569" type="indirect"></relation>
</listRelation>
<tutelles><tutelle active="#struct-2496" type="direct"><org type="laboratory" xml:id="struct-2496" status="OLD"> <orgName>INRIA Lorraine</orgName>
<desc> <address> <addrLine>615 rue du Jardin Botanique 54600 Villers-lès-Nancy</addrLine>
<country key="FR"></country>
</address>
<ref type="url">http://www.inria.fr/centre-de-recherche-inria/nancy-grand-est</ref>
</desc>
<listRelation> <relation active="#struct-300009" type="direct"></relation>
</listRelation>
</org>
</tutelle>
<tutelle active="#struct-300009" type="indirect"><org type="institution" xml:id="struct-300009" status="VALID"> <orgName>Institut National de Recherche en Informatique et en Automatique</orgName>
<orgName type="acronym">Inria</orgName>
<desc> <address> <addrLine>Domaine de VoluceauRocquencourt - BP 10578153 Le Chesnay Cedex</addrLine>
<country key="FR"></country>
</address>
<ref type="url">http://www.inria.fr/en/</ref>
</desc>
</org>
</tutelle>
<tutelle active="#struct-466633" type="direct"><org type="laboratory" xml:id="struct-466633" status="OLD"> <orgName>Laboratoire Lorrain de Recherche en Informatique et ses Applications</orgName>
<orgName type="acronym">LORIA</orgName>
<desc> <address> <addrLine>Campus Scientifique BP 239 54506 Vandoeuvre-lès-Nancy Cedex</addrLine>
<country key="FR"></country>
</address>
<ref type="url">http://www.loria.fr</ref>
</desc>
<listRelation> <relation active="#struct-300009" type="direct"></relation>
<relation active="#struct-300291" type="direct"></relation>
<relation active="#struct-300292" type="direct"></relation>
<relation active="#struct-300293" type="direct"></relation>
<relation name="UMR7503" active="#struct-441569" type="direct"></relation>
</listRelation>
</org>
</tutelle>
<tutelle active="#struct-300291" type="indirect"><org type="institution" xml:id="struct-300291" status="OLD"> <orgName>Université Henri Poincaré - Nancy 1</orgName>
<orgName type="acronym">UHP</orgName>
<date type="end">2011-12-31</date>
<desc> <address> <addrLine>24-30 rue Lionnois, BP 60120, 54 003 NANCY cedex, France</addrLine>
<country key="FR"></country>
</address>
</desc>
</org>
</tutelle>
<tutelle active="#struct-300292" type="indirect"><org type="institution" xml:id="struct-300292" status="OLD"> <orgName>Université Nancy 2</orgName>
<date type="end">2011-12-31</date>
<desc> <address> <addrLine>91 avenue de la Libération, BP 454, 54001 Nancy cedex</addrLine>
<country key="FR"></country>
</address>
</desc>
</org>
</tutelle>
<tutelle active="#struct-300293" type="indirect"><org type="institution" xml:id="struct-300293" status="OLD"> <orgName>Institut National Polytechnique de Lorraine</orgName>
<orgName type="acronym">INPL</orgName>
<date type="end">2011-12-31</date>
<desc> <address> <country key="FR"></country>
</address>
</desc>
</org>
</tutelle>
<tutelle name="UMR7503" active="#struct-441569" type="indirect"><org type="institution" xml:id="struct-441569" status="VALID"> <idno type="IdRef">02636817X</idno>
<idno type="ISNI">0000000122597504</idno>
<orgName>Centre National de la Recherche Scientifique</orgName>
<orgName type="acronym">CNRS</orgName>
<date type="start">1939-10-19</date>
<desc> <address> <country key="FR"></country>
</address>
<ref type="url">http://www.cnrs.fr/</ref>
</desc>
</org>
</tutelle>
</tutelles>
</hal:affiliation>
<country>France</country>
<placeName><settlement type="city">Nancy</settlement>
<region type="region" nuts="2">Grand Est</region>
<region type="old region" nuts="2">Lorraine (région)</region>
</placeName>
<orgName type="university">Université Nancy 2</orgName>
<orgName type="institution" wicri:auto="newGroup">Université de Lorraine</orgName>
<placeName><settlement type="city">Nancy</settlement>
<region type="region" nuts="2">Grand Est</region>
<region type="old region" nuts="2">Lorraine (région)</region>
</placeName>
<orgName type="university">Institut national polytechnique de Lorraine</orgName>
<orgName type="institution" wicri:auto="newGroup">Université de Lorraine</orgName>
</affiliation>
</author>
</titleStmt>
<publicationStmt><idno type="wicri:source">HAL</idno>
<idno type="RBID">Hal:inria-00098462</idno>
<idno type="halId">inria-00098462</idno>
<idno type="halUri">https://hal.inria.fr/inria-00098462</idno>
<idno type="url">https://hal.inria.fr/inria-00098462</idno>
<date when="1998">1998</date>
<idno type="wicri:Area/Hal/Corpus">000037</idno>
<idno type="wicri:Area/Hal/Curation">000037</idno>
<idno type="wicri:Area/Hal/Checkpoint">000031</idno>
<idno type="wicri:explorRef" wicri:stream="Hal" wicri:step="Checkpoint">000031</idno>
<idno type="wicri:Area/Main/Merge">002603</idno>
<idno type="wicri:Area/Main/Curation">002483</idno>
<idno type="wicri:Area/Main/Exploration">002483</idno>
<idno type="wicri:Area/France/Extraction">000227</idno>
</publicationStmt>
<sourceDesc><biblStruct><analytic><title xml:lang="fr">Noms propres, syntagmes nominaux, expressions référentielles : repérage et codage.</title>
<author><name sortKey="Bruneseaux, Florence" sort="Bruneseaux, Florence" uniqKey="Bruneseaux F" first="Florence" last="Bruneseaux">Florence Bruneseaux</name>
<affiliation wicri:level="1"><hal:affiliation type="researchteam" xml:id="struct-2351" status="OLD"> <idno type="RNSR">199421391G</idno>
<orgName>Human-machine dialogue with a significant language component</orgName>
<orgName type="acronym">LANGUE ET DIALOGUE</orgName>
<desc> <address> <country key="FR"></country>
</address>
</desc>
<listRelation> <relation active="#struct-2496" type="direct"></relation>
<relation active="#struct-300009" type="indirect"></relation>
<relation active="#struct-466633" type="direct"></relation>
<relation active="#struct-300291" type="indirect"></relation>
<relation active="#struct-300292" type="indirect"></relation>
<relation active="#struct-300293" type="indirect"></relation>
<relation name="UMR7503" active="#struct-441569" type="indirect"></relation>
</listRelation>
<tutelles><tutelle active="#struct-2496" type="direct"><org type="laboratory" xml:id="struct-2496" status="OLD"> <orgName>INRIA Lorraine</orgName>
<desc> <address> <addrLine>615 rue du Jardin Botanique 54600 Villers-lès-Nancy</addrLine>
<country key="FR"></country>
</address>
<ref type="url">http://www.inria.fr/centre-de-recherche-inria/nancy-grand-est</ref>
</desc>
<listRelation> <relation active="#struct-300009" type="direct"></relation>
</listRelation>
</org>
</tutelle>
<tutelle active="#struct-300009" type="indirect"><org type="institution" xml:id="struct-300009" status="VALID"> <orgName>Institut National de Recherche en Informatique et en Automatique</orgName>
<orgName type="acronym">Inria</orgName>
<desc> <address> <addrLine>Domaine de VoluceauRocquencourt - BP 10578153 Le Chesnay Cedex</addrLine>
<country key="FR"></country>
</address>
<ref type="url">http://www.inria.fr/en/</ref>
</desc>
</org>
</tutelle>
<tutelle active="#struct-466633" type="direct"><org type="laboratory" xml:id="struct-466633" status="OLD"> <orgName>Laboratoire Lorrain de Recherche en Informatique et ses Applications</orgName>
<orgName type="acronym">LORIA</orgName>
<desc> <address> <addrLine>Campus Scientifique BP 239 54506 Vandoeuvre-lès-Nancy Cedex</addrLine>
<country key="FR"></country>
</address>
<ref type="url">http://www.loria.fr</ref>
</desc>
<listRelation> <relation active="#struct-300009" type="direct"></relation>
<relation active="#struct-300291" type="direct"></relation>
<relation active="#struct-300292" type="direct"></relation>
<relation active="#struct-300293" type="direct"></relation>
<relation name="UMR7503" active="#struct-441569" type="direct"></relation>
</listRelation>
</org>
</tutelle>
<tutelle active="#struct-300291" type="indirect"><org type="institution" xml:id="struct-300291" status="OLD"> <orgName>Université Henri Poincaré - Nancy 1</orgName>
<orgName type="acronym">UHP</orgName>
<date type="end">2011-12-31</date>
<desc> <address> <addrLine>24-30 rue Lionnois, BP 60120, 54 003 NANCY cedex, France</addrLine>
<country key="FR"></country>
</address>
</desc>
</org>
</tutelle>
<tutelle active="#struct-300292" type="indirect"><org type="institution" xml:id="struct-300292" status="OLD"> <orgName>Université Nancy 2</orgName>
<date type="end">2011-12-31</date>
<desc> <address> <addrLine>91 avenue de la Libération, BP 454, 54001 Nancy cedex</addrLine>
<country key="FR"></country>
</address>
</desc>
</org>
</tutelle>
<tutelle active="#struct-300293" type="indirect"><org type="institution" xml:id="struct-300293" status="OLD"> <orgName>Institut National Polytechnique de Lorraine</orgName>
<orgName type="acronym">INPL</orgName>
<date type="end">2011-12-31</date>
<desc> <address> <country key="FR"></country>
</address>
</desc>
</org>
</tutelle>
<tutelle name="UMR7503" active="#struct-441569" type="indirect"><org type="institution" xml:id="struct-441569" status="VALID"> <idno type="IdRef">02636817X</idno>
<idno type="ISNI">0000000122597504</idno>
<orgName>Centre National de la Recherche Scientifique</orgName>
<orgName type="acronym">CNRS</orgName>
<date type="start">1939-10-19</date>
<desc> <address> <country key="FR"></country>
</address>
<ref type="url">http://www.cnrs.fr/</ref>
</desc>
</org>
</tutelle>
</tutelles>
</hal:affiliation>
<country>France</country>
<placeName><settlement type="city">Nancy</settlement>
<region type="region" nuts="2">Grand Est</region>
<region type="old region" nuts="2">Lorraine (région)</region>
</placeName>
<orgName type="university">Université Nancy 2</orgName>
<orgName type="institution" wicri:auto="newGroup">Université de Lorraine</orgName>
<placeName><settlement type="city">Nancy</settlement>
<region type="region" nuts="2">Grand Est</region>
<region type="old region" nuts="2">Lorraine (région)</region>
</placeName>
<orgName type="university">Institut national polytechnique de Lorraine</orgName>
<orgName type="institution" wicri:auto="newGroup">Université de Lorraine</orgName>
</affiliation>
</author>
</analytic>
</biblStruct>
</sourceDesc>
</fileDesc>
<profileDesc><textClass><keywords scheme="mix" xml:lang="it"><term>annotation linguistique</term>
<term>linguistic annotation</term>
<term>name</term>
<term>nom</term>
<term>référence</term>
<term>sgml</term>
<term>standardisation</term>
<term>standardization</term>
<term>tei</term>
</keywords>
</textClass>
</profileDesc>
</teiHeader>
<front><div type="abstract" xml:lang="fr">Parmi les avantages qu'offre la version informatisée d'une ressource linguistique, il y a, entre autres, la possibilité d'enrichir le document d'annotations spécifiques qui ne se limitent pas à un simple repérage de début/fin de sections ou de paragraphes. Dans cet article, nous aborderons plus précisément le problème du repérage et du codage des noms propres, syntagmes nominaux et expressions référentielles. Cependant, si l'annotation des noms propres peut être intéressante à des fins multiples (résumés automatiques, recherche dans des bases de données, etc.), on verra que dans les faits un tel travail suppose une bonne réflexion sur ce que l'on doit effectivement coder. C'est pourquoi, en nous appuyant sur les recommandations de la TEI (Text Encoding Initiative), nous faisons des propositions afin d'aller au-delà des possibilités actuelles et d'offrir ainsi un schéma qui permette d'affiner le codage en fonction du niveau d'analyse auquel le nom propre est appréhendé, distinguant entre nom propre élément d'un syntagme nominal ou d'une expression référentielle. || Among the advantages of an electronic version of a document is the oportunity to include different kinds of annotations which are not restricted to section or paragraph tagging. This paper discusses the encoding of proper names, nominal phrases and referr</div>
</front>
</TEI>
<affiliations><list><country><li>France</li>
</country>
<region><li>Grand Est</li>
<li>Lorraine (région)</li>
</region>
<settlement><li>Nancy</li>
</settlement>
<orgName><li>Institut national polytechnique de Lorraine</li>
<li>Université Nancy 2</li>
<li>Université de Lorraine</li>
</orgName>
</list>
<tree><country name="France"><region name="Grand Est"><name sortKey="Bruneseaux, Florence" sort="Bruneseaux, Florence" uniqKey="Bruneseaux F" first="Florence" last="Bruneseaux">Florence Bruneseaux</name>
</region>
</country>
</tree>
</affiliations>
</record>
Pour manipuler ce document sous Unix (Dilib)
EXPLOR_STEP=$WICRI_ROOT/Wicri/Informatique/explor/SgmlV1/Data/France/Analysis
HfdSelect -h $EXPLOR_STEP/biblio.hfd -nk 000227 | SxmlIndent | more
Ou
HfdSelect -h $EXPLOR_AREA/Data/France/Analysis/biblio.hfd -nk 000227 | SxmlIndent | more
Pour mettre un lien sur cette page dans le réseau Wicri
{{Explor lien |wiki= Wicri/Informatique |area= SgmlV1 |flux= France |étape= Analysis |type= RBID |clé= Hal:inria-00098462 |texte= Noms propres, syntagmes nominaux, expressions référentielles : repérage et codage. }}
This area was generated with Dilib version V0.6.33. |